AI资讯新闻榜单内容搜索- Agent

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索:  Agent
更可信、更省钱的Agent?实测OpenSquilla

更可信、更省钱的Agent?实测OpenSquilla

更可信、更省钱的Agent?实测OpenSquilla

上周有个项目,让我觉得很有意思。GitHub上一个叫OpenSquilla的,发布不到一个月,Star涨到了5300多。OpenSquilla 0.4.0,定位Token-Efficient AI Agent,是一个很有效率又很有创意的智能体框架。

来自主题: AI技术研报
10180 点击    2026-07-06 19:34
Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

为了解决这一问题,来自 University of Arizona、Zoom 与 Stony Brook University 的研究团队推出了 VISTA(VIsual Spec-To-App Benchmark), 首个面向 Visual Spec-to-Web-App Coding Agents 的端到端 Benchmark。

来自主题: AI技术研报
8521 点击    2026-07-06 15:49
Claude Code用不了?DeepSeek上新:Deep Code来了

Claude Code用不了?DeepSeek上新:Deep Code来了

Claude Code用不了?DeepSeek上新:Deep Code来了

据DeepSeek官方API文档及GitHub仓库信息,一款名为Deep Code的第三方开源AI编程助手近日被收录进DeepSeek Agent工具。该工具面向DeepSeek-V4系列模型做了适配,支持深度思考、推理强度控制、Agent Skills以及MCP集成。截至发稿,Deep Code GitHub仓库显示,该工具收获超1500星、127 fork。

来自主题: AI资讯
9095 点击    2026-07-06 14:40
一群 AI Native 创始人,正在长出来

一群 AI Native 创始人,正在长出来

一群 AI Native 创始人,正在长出来

这几天,我们把一群平均年龄只有 19 岁的人召集到一起。几天之后,我们意识到,这可能是一次提前到来的未来。他们来自不同地方,有人做模型、做 agent、做机器人,有人做硬件、做开发者工具,有人还在上学,有人则已经在真实产品里承担核心工作。这里面有一批人已经站在今天 AI 最前沿的地方,参与过很多人正在使用、讨论、追赶的基座模型。

来自主题: AI资讯
7996 点击    2026-07-06 10:46
vercel-labs/skills 狂揽2.4万星标:一行命令,AI会自己找技能了

vercel-labs/skills 狂揽2.4万星标:一行命令,AI会自己找技能了

vercel-labs/skills 狂揽2.4万星标:一行命令,AI会自己找技能了

这个官方仓库vercel-labs/skills,发布仅五个月,GitHub星标就冲到了2.4万。凭什么这么火?简单到只有一行命令:npx skills add <package>。说白了,它就是AI智能体(AI agent)的包管理器。

来自主题: AI资讯
10616 点击    2026-07-06 10:41
把 Kimi 接进 Codex ,小白用 Agent 的最好选择

把 Kimi 接进 Codex ,小白用 Agent 的最好选择

把 Kimi 接进 Codex ,小白用 Agent 的最好选择

如果是小白第一次上手,我会更建议从 Kimi 开始。Kimi 的中文理解、长文本处理、Coding、多模态综合能力都很强,是最适合 Codex 的国产模型。今天这篇内容,手把手教大家如何将第三方大模型接入 Codex 搞定日常任务。

来自主题: AI资讯
10837 点击    2026-07-05 11:05
Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

Router的作用被低估了?vLLM这个神器,让单次调用背后藏了一支模型协作小队

vLLM 社区推出的 Semantic Router 除了专注上面三个方向,正在更进一步:我们认为:router 不只是选择模型,还可以提升模型能力。用户不用改权重,也不用让每个 Agent 团队都自己搭一套 Graph,而是在一次普通 Model API 调用的内部,组织出一支有边界、有预算、有验证、有回退的 “小队”。

来自主题: AI技术研报
9166 点击    2026-07-05 09:43
把Agent丢入1000+文件:人大CoDA-Bench揭示Code Agent瓶颈

把Agent丢入1000+文件:人大CoDA-Bench揭示Code Agent瓶颈

把Agent丢入1000+文件:人大CoDA-Bench揭示Code Agent瓶颈

中国人民大学的研究团队提出 CoDA-Bench,联合评估 Agent 的 Code Intelligence + Data Intelligence。该基准首次把 Code Agent 放进包含 1000 + 数据文件的复杂环境下,要求模型先自主探索文件系统、找到相关数据,再编写代码完成分析。实验显示,即使当前表现最好的系统,在 CoDA-Bench 上执行准确率也只有 61.1%;

来自主题: AI技术研报
9689 点击    2026-07-04 10:51
AI Agent为什么总是不稳定?终于有了一个系统性基准来拆解

AI Agent为什么总是不稳定?终于有了一个系统性基准来拆解

AI Agent为什么总是不稳定?终于有了一个系统性基准来拆解

三星大模型团队联合北京大学、香港城市大学、香港科技大学等科研机构,共同发布了面向 AI Agent 的基准测试 LiveClawBench。它关注的并不是「谁的 Agent 更强」,而是一个更基础、也更关键的问题:为什么同一个 AI Agent,在一些任务中已经接近可用,而在另一些任务中却会突然失稳?

来自主题: AI技术研报
7855 点击    2026-07-04 10:50
今天刚听完的硅谷 AI 工程师实践分享:AI agent 到底怎么才算真正落地

今天刚听完的硅谷 AI 工程师实践分享:AI agent 到底怎么才算真正落地

今天刚听完的硅谷 AI 工程师实践分享:AI agent 到底怎么才算真正落地

今晚,我在旧金山 Howard Street 的 Inngest 总部,参加了一场叫做 {AI} in Production 的小型聚会。主办方是 Inngest,Cursor、Arcade、Vapi 联合参与。清一色是在一线真正跑 AI agent 的工程师和创始人,一群人坐在一起,讲他们把 AI 部署进生产环境之后遇到的真实问题。

来自主题: AI资讯
9223 点击    2026-07-03 16:13